Skip to content
  • 0 Votes
    1 Posts
    96 Views
    A
    <p>Nach den neuesten Abrechnungsregeln von OpenAI verwenden Modelle wie GPT-5.6 Sol für Anfragen mit extrem langen Kontexten eine gestaffelte Preisstruktur.</p><p>Wenn der Kontext einer einzelnen Anfrage 272K Tokens überschreitet, können Eingabe, Cache-Lesevorgänge und Ausgabe nach einer höheren Preisstufe abgerechnet werden. Diese Regel stammt aus der offiziellen Preisgestaltung von OpenAI und stellt weder einen vorübergehenden Aufschlag noch eine fehlerhafte Abrechnung durch AI-ROUTER dar.</p><p></p><p>Am Beispiel der Standardpreise für GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Position Bis 272K Über 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Eingabe $5 / 1M Tokens $10 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache-Lesevorgänge $0.50 / 1M Tokens $1 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ausgabe $30 / 1M Tokens $45 / 1M Tokens</code></pre><p></p><p>Die endgültigen Kosten werden weiterhin anhand der jeweiligen Gruppe, des Kontomultiplikators und anderer Abrechnungseinstellungen berechnet.</p><p></p><p>Das x2-Kennzeichen in den Nutzungsdaten bedeutet, dass diese Anfrage die gestaffelte Abrechnung für lange Kontexte ausgelöst hat. Das Kennzeichen weist hauptsächlich darauf hin, dass Eingabe und Cache-Lesevorgänge in eine höhere Preisstufe fallen. Es bedeutet nicht, dass sich alle Kosten der gesamten Anfrage einfach verdoppeln; für die Ausgabe kann ein anderer Staffelmultiplikator gelten.</p><p></p><p><strong> ## So vermeiden Sie die gestaffelte Abrechnung</strong></p><p>Wenn kein Kontextfenster mit 1M Tokens benötigt wird, empfiehlt es sich, das Codex-Kontextlimit wieder auf höchstens 272K zu setzen.</p><p></p><p>Öffnen Sie:</p><p> ~/.codex/config.toml</p><p></p><p>Ändern Sie die ursprüngliche Konfiguration für 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>zu:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Speichern Sie die Datei, starten Sie Codex neu und beginnen Sie eine neue Sitzung.</p><p></p><p>Wenn die Änderung nur vorübergehend für eine einzelne Sitzung gelten soll, können Sie Folgendes verwenden:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zusätzlich wird empfohlen:</p><p> - die automatische Komprimierung rechtzeitig zu aktivieren;</p><p> - besonders lange Aufgaben auf mehrere Sitzungen aufzuteilen;</p><p> - die Menge der auf einmal zurückgegebenen Tool-Ausgaben zu reduzieren;</p><p> - frühere Gesprächsinhalte regelmäßig zusammenzufassen und zu bereinigen.</p><p></p><p>Wenn tatsächlich ein Kontextfenster mit 1M Tokens benötigt wird, kann die ursprüngliche Konfiguration weiterhin verwendet werden. Nach Überschreiten von 272K werden jedoch die höheren Preisstufen von OpenAI berechnet.</p><p></p><p>Eine Beschreibung der ursprünglichen Konfiguration finden Sie unter: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">So aktivieren Sie in Codex ein Kontextfenster mit 1 Million Tokens für GPT-5.6 Sol </a></p><p></p><p>Vielen Dank für Ihr Verständnis und Ihre Unterstützung.</p>